第 09 章 · 第三步:指挥 AI 干活

第09章 自动运营:任务、轮次与验收

把任务交给 AI 之后,它到底是怎么"排班干活"的?这一章带你看懂任务、时间片、轮次、重排、验收和人工节点——全书最核心的一章。

阅读约 35 分钟 新手友好 重点:排班与验收 附 5 个附录

前面几章你已经完成了三件事:建好了公司、创建了项目、给项目配好了运行模式和预算(第 04 章),甚至已经通过智能体中心建好了几个 AI 员工(第 08 章)。现在,你站在整个平台最关键的一道门前——让 AI 真正开始"上班"。

很多新手的直觉是:给 AI 下一条大指令,等它几天后交活。真跑起来你会发现完全不是这样。AI 需要一套排班制度:谁先干、干多久、干完怎么交接、干砸了怎么办、钱不够了怎么刹车。这套制度,就是本产品里最硬核、也最值钱的一块能力——自动运营(英文叫 auto-ops)。

一个贯穿全章的比喻:AI 小工厂的排班表

把项目想象成一家 24 小时开工的小工厂。厂里有几台机床(任务),有一张挂在墙上的排班表(时间片),工人每上一"班"就照表干活(轮次)。每班结束,工头会把"这班干了啥、还剩啥"写进交接本(任务接力),下一班接着干。干完一件活,不能自己说"我干好了",得交给独立质检员(验收)。遇到要老板签字的活(人工处理节点),就贴张单子等你。厂子空了就"待工省电"(空闲等待)。钱快花超了就拉闸(预算熔断)。

这一章,我们就把这张排班表从里到外看一遍。看完你就能既让 AI 高效干活,又不会让它瞎烧钱。

你将学会

一、自动运营控制台:你的工厂总控室

自动运营控制台是这套机制的"仪表盘+总开关"。所有关于排班、预算、状态的实时信息,都汇聚在这一页。

进入项目 › 左侧菜单「组织与运营」 › 自动运营

1.1 顶部的六个按钮

打开控制台,最上方一排按钮就是你的"总开关"。它们的含义如下:

按钮点下去会发生什么什么时候用
启动为这个项目拉起独立的自动运营循环,AI 开始按排班表干活项目刚配好,或暂停后要重新开工
暂停发出暂停信号,当前这一轮跑完才进入等待(不打断正在干活的子进程,避免丢上下文)临时要改方向、要开会、暂时不想让它跑
恢复从下一轮继续,保留已有排班和任务接力信息暂停后想接着原来的进度干
停止停止循环并强停当前轮,状态置为「已停止」,服务重启也不会自动拉起这个项目暂时封存,不想它再自动跑
终止项目把项目置为"终止态",并生成一份结项报告项目做完了、或决定彻底不做了
刷新重新拉取当前页数据想立刻看到最新状态

另外左上角还有一个 返回项目,回到项目主页。这几个按钮都会弹确认框,其中「停止」的确认文案是——

界面原文 · 停止确认 确定停止自动运营?此操作不可撤销

而「终止项目」会弹一个输入框,提示:请输入终止原因(将置终止态并生成结项报告)。终止是不可逆的,想清楚再点。

暂停 ≠ 停止,别点错

暂停是"先歇一会儿",循环还在,随时能「恢复」;停止是"收工",服务重启都不会自己跑起来,要重新「启动」。日常临时改东西用暂停,长期不跑用停止。

1.2 四张状态卡片

按钮下方是四张卡片,一眼看清项目"现在什么状态、花了多少钱":

运行模式

显示当前是全自动、半自动还是人工审核。旁边有 修改 按钮,点开可临时调整。

自主级别

显示 L0~L3,默认 L2。级别越高,AI 越自由(详见第七章)。

任务数

这个项目当前登记了多少任务。

累计花费

项目至今的累计花费金额,是红色高亮显示的。

1.3 "AI 预算消耗"卡:钱花到哪一步了

再往下是预算区。这里会显示一行文字:

界面原文 · 预算消耗 本轮预算: ¥100.00 / 已用 ¥12.30

当用量百分比达到预警线时,这里会出现一个琥珀色的「预警」标签,提醒你该考虑补充预算了。预警线由后端统一下发(默认 80%,卡片上会直接标出「预警线 N%」),和「计费明细」页是同一套口径,不会出现两个页面各说各话。

1.4 "预算运行态"卡:三道保险的实时状态

这一张卡片把三种"防烧钱保险"的状态并排显示:

标签含义
熔断:是 / 否"是"表示预算已耗尽,循环被自动拉闸暂停
降级:是 / 否"是"表示系统正以降级模式运行(如模型/引擎降档以省成本)
已终止:是 / 否"是"表示项目已进入终止态

卡片底部还会显示"总预算 ¥x / 已用 ¥y · AI ¥x / 已用 ¥y",把总预算和AI 运行预算两条线分开列清楚。

1.5 "项目已因兜底保护暂停"——最关键的一条报警

如果系统因为连续失败或预算问题自动刹车了,控制台顶部会出现一条醒目的告警,标题是:

界面原文 · 兜底保护告警 项目已因兜底保护暂停
原因:…… · 暂停时间:……
兜底暂停为持久状态(跨重启保留),需人工在运行配置 / 任务面板处理后,点击「恢复」继续。
这条告警不会自己消失

兜底暂停是持久状态——就算你把项目服务器重启,它还是暂停的。这是故意的:出问题时必须由人去看一眼、处理掉根因,再手动点「恢复」。不处理就点恢复,很可能下一轮又立刻被刹停。

另外注意:处在这种状态时,顶部状态标签会显示「已暂停(兜底)」,不会再挂着绿色的「运行中」——别被一个绿标签骗过去,以为它还在正常干活。

1.6 十六个快捷入口

控制台下方排着一整屏快捷入口,它们是本章后面各节的入口,也是你日常最常点的位置(顺序如下):

任务管理 · 运行轮次 · 日志面板 · 计费明细 · 人工节点 · 角色管理 · 目标管理 · 审计治理 · 经营日报 · 监控指标 · 结项报告 · 验收记录 · 测试运行 · 阿米巴核算 · 经营驾驶舱 · 权限租赁

新手只要先记住四个

任务管理(我要 AI 干啥)、运行轮次(AI 现在干到哪了)、人工节点(有没有等我点确认的)、计费明细(花了多少钱)。其余入口用到再点,本章后面会逐个讲。

1.7 改运行模式:全自动 / 半自动 / 人工审核

点运行模式卡片旁的「修改」,会弹出「调整运行模式与预算科目」窗口。三个选项及其官方说明如下:

选项界面上给你的说明(原文)
全自动AI 自动拆解任务、调度轮次、评审验收,全程自动执行,仅在关键节点通知你。
半自动AI 自动执行,但在关键决策节点(目标变更、大额支出、对外动作等)由人工确认后继续。
人工审核AI 产出方案后必须人工审核通过才执行,节奏较慢但最可控。

选到「人工审核」时,界面上会出现一条提醒:

界面原文 · 人工审核提醒 切换后将暂停自动运营循环,仅保留人工审核驱动的执行,可在之后重新启动或调整
只有"全自动 / 半自动"会真的自己跑

请记住:只有全自动和半自动模式会启用自动运营循环;切到「人工审核」后,循环会暂停,任务要靠你手动触发。另外,在创建项目向导里这个选项叫「手动」,进了项目控制台后叫「人工审核」,它们是同一个东西。

同一个窗口里还能调整"预算科目"(把 AI 的花费归到哪个科目)。界面提示:常用科目:token_fee(模型调用)/ third_party_api(第三方接口)/ compute_fee(算力)/ human_intervention(人工介入),留空科目将不计入。

二、任务:给工厂安排机床

工厂要开工,先得有活干。"任务"就是一件件要被 AI 完成的活。它是整个自动运营的基本单位——后面讲的时间片、轮次、验收、计费,全都围绕任务展开。

自动运营控制台 › 任务管理

2.1 任务列表长什么样

进入「任务管理」,右上角有 新建任务。列表顶部有六个筛选标签,点一下就能只看某一类任务:待执行 / 运行中 / 已暂停 / 已完成 / 失败 / 规划中。

表格的列依次是:任务名称 / 状态 / 优先级 / 时间片 / 引擎 / 类型 / 模型 / 创建时间 / 操作。其中"模型"列如果没单独指定,会统一显示「路由自动」——意思是交给平台的模型网关自己挑合适的模型。

每一行的"操作"区最多会出现这几个按钮:编辑、继续规划(软件工程类处于规划中时)、继续修改(软件修改类处于规划中时)、查看规划(软件工程类已提交执行后,只读回看)、恢复(暂停时)、暂停(运行时)、删除(仅规划中)。

只有"规划中"的任务可以删除

任务列表里,处于「规划中」的任务(也就是软件工程/软件修改建好但还没走完向导的那些)操作区会多出一个 删除 按钮,点了会先弹二次确认。这是给你清理"中途放弃的向导任务"用的。

反过来,已经进入待执行 / 运行中 / 已完成的任务不可删除——点了接口会返回 400 并说明原因。想让一个正在跑的任务不再执行,稳妥做法是暂停它,或编辑它的提示词模板把方向改掉,等下一次 review 重排。这样设计是为了防止误删正在推进或已验收留痕的任务。

2.2 新建任务时,每个字段怎么填

点 新建任务,弹窗里字段不少,但真正需要你想清楚的只有四五个。逐个说明:

字段怎么理解 / 怎么填
任务名称(必填)一句话说清干什么,例如 placeholder 里给的示例:如:市场定向调研。别写"任务1"这种没信息量的名字。
描述(必填,最多 500 字)把要求写具体。特别重要:请把"什么样算做完"也写进这里(原因见 2.4)。
任务类型三选一:通用任务 / 新建软件工程 / 软件修改。后两类会走软件工程专用流程(详见第 10 章)。
软件名称只有"新建软件工程"才出现。留空则自动命名(按任务标题或序号)。填了它,这个软件的 PRD/TAD/模块文档就会写进独立的子目录,和项目里别的软件互不覆盖(详见第 10 章)。
优先级P0-紧急 / P1-高 / P2-常规 / P3-低。用来决定该任务在排班中的轻重。
时间片权重1~10,默认 1。这是分配精力的旋钮:权重越高,每轮分给它的时间片越多。详见第三章。创建后不可修改。
引擎类型循环执行(loop)适合复杂、编码、长时任务;Agent 智能体(Agent 引擎)适合信息整合、接口调用、快速任务。
AI 模型留空即「路由自动」,由网关按任务复杂度挑模型。
关联软件工程仅"软件修改"类任务需要选。
时限(秒)默认 7200 秒(2 小时),步进 60。单轮超过这个时长会被强杀,防止无限运行。
角色 ID可选。placeholder:指派 Agent 角色 ID(可选)。指定后由这个 AI 员工来干。
提示词模板可选。placeholder:任务执行提示词模板。想固定 AI 的干活套路时填。
哪些字段建好之后还能改?

在任务列表点「编辑」时,弹窗顶部会明确告诉你能改什么:可改——优先级、引擎类型、时限、AI 模型、提示词模板;不可改——任务名称、任务描述、时间片权重、角色 ID。

为什么把描述锁死?因为描述是独立验收 Agent 的对照依据(验收要拿"当初说好什么算做完"来判),中途改描述等于换了尺子。所以请一次就把"什么算做完"写清楚。补充或纠偏信息的正确出口是:编辑任务的描述(首次填写时)或任务级提示词模板——界面上没有独立的"注入信息"按钮,别找。

另外,编辑时「时限(秒)」留空表示保持原值,不会被悄悄重置成默认的 7200。

2.3 引擎怎么选:一个警示弹窗救了很多人

如果你选了"新建软件工程 / 软件修改"这类任务类型,却把引擎选成了 Agent 智能体,界面会弹出一条警告:

界面原文 · 引擎选择警告 Agent 引擎可能无法完成软件交付,仅适合简单项目,建议使用循环执行
要交付软件,就用"循环执行"

两条经验:要写代码、做工程、跑长任务的,选「循环执行」;只是查资料、做汇总、调接口的短活,选「Agent 智能体」。不指定时,系统会根据描述里的关键词自动猜(编码/开发/构建→循环;查询/汇总/快速→Agent;拿不准→循环)。引擎的最终优先级是:任务级 > 角色级 > 项目默认。

2.4 界面没有"验收标准"输入框,怎么办?

这是新手最容易踩的一个坑,务必看清:当前界面并没有一个独立的"验收标准"输入框(这个字段在系统接口层是存在的,只是暂时没有放到界面上)。所以,

这样做:把"什么算做完"直接写进任务描述里。例如:

产出 3 篇 B2B 英文邮件文案,每篇含主题行、正文、CTA 按钮文案,并通过事实自检。

别这样做:只写"写几篇营销文案"就提交。AI 不知道做到什么程度算达标,容易提前宣布完成,或反复返工。

写点营销文案。 ✗

判定任务"完成"的硬信号,是 AI 在输出末尾打出 `[Task finished]` 标记(详见第六章)。而它判断自己达没达标,依据就是你在描述里写的标准。所以,描述写得多清楚,AI 就干得多靠谱。

2.5 中途想补充信息怎么办

项目跑起来后,你常常会想补充需求,比如"客户要求周三前交付"。系统里"注入新信息"的说法确实存在,在你看到的那条空闲等待消息里也会出现。但要先明确一条规则:自动运营任务的「描述」创建后不可修改(它是独立验收的对照依据)。所以补充信息的可行路径是:

  1. 在任务列表找到那条任务,点 编辑;
  2. 把新信息写进任务级「提示词模板」(不要试图改描述,编辑态下它是只读的);
  3. 保存。下一轮调度到它时,AI 就会看到更新后的提示词。

如果改动大到连目标都变了,更干净的做法是新建一个任务,让旧任务走完或被暂停。

另外,如果你用的是"智能体"里的 Agent 任务(第 08 章),那个页面有一个专门的 注入 按钮,可以在任务运行中实时投喂信息。两者不要混淆:自动运营任务靠"编辑描述",Agent 任务靠"注入信息"。

三、时间片与轮次:排班表怎么转起来

这是本章最"硬核"的一节,但只要抓住一个比喻就好懂:排班表上有 10 个格子(时间片),工人每上一班(一轮)就照表做一个格子的活。

3.1 10 个时间片,任务按权重"占格子"

系统默认把调度表切成 10 个时间片。每个任务按它的时间片权重(1~10)去"占格子":

所以"时间片权重"本质上是你给它分配的精力比例。重要的、要尽快出结果的活,权重调高;日常维护类的小活,权重给 1 就行。

任务多了,格子会自动扩容

如果未完成任务的权重加起来超过了 10,系统会自动把格子扩到够用,保证没有任务会被"漏掉"。你不需要手动算格子数。

3.2 一轮 = 一个格子的活

每推进一个时间片,就产生一次轮次(round)。轮次是整个自动运营的"心跳"。轮到某个任务时,系统会:

  1. 把它上一轮留下的任务接力信息注入提示词(见 3.3);
  2. 调用引擎真的去干活(跑代码、调模型、调接口);
  3. 把这一轮的执行记录、耗时、花费、日志都落下来;
  4. 判断这一轮的产出是否出现了完成标记。

轮次分三种模式,你在「运行轮次」页面的"模式"列能看到:

模式叫什么干什么
task任务轮按排班表挑一个未完成任务,干一个时间片的活
reviewreview 轮让 AI 抬头看全局,重排任务与时间片(见第四章)
free空闲等待轮没活可干时待工省电,只做常规检查(见第五章)

3.3 任务接力:AI 为什么能"接着上一轮继续干"

这是很多新手最好奇的点:AI 又没有记忆,凭什么下一轮能接着上轮干?答案是——每轮结束时,系统会让它写一张"交接条",内容包括:

这张交接条会保存下来,下一轮轮到同一个任务时,自动注入提示词。AI 就像工人翻开上一班的交接本,照着"下一步"接着干。这个机制,读起来像是"接力棒",所以本手册统一叫它任务接力。

接力信息是"过程记忆",不是"结果报告"

接力信息记录的是进度(干到哪、下一步干啥),不是验收结论。任务的最终结论由独立验收 Agent 给出(第六章)。这也是为什么"完成"必须靠硬标记——光靠接力说"快好了"是不算数的。

3.4 怎么看 AI 干到哪了:运行轮次页

自动运营控制台 › 运行轮次

页面标题是「运行轮次与日志」,表格列有:轮次 / 状态 / 模式 / 引擎 / 耗时(秒)/ 花费(元)/ 开始时间。你可以一眼看到每一轮干得好不好、花了多少钱。

"状态"列的取值有:待执行 / 运行中 / 已通过 / 需重做 / 已驳回 / 失败。后三个(需重做、已驳回、失败)出现时就要留意了,说明这一轮没过关或出了问题。

点开任意一轮,可以看它的实时日志:

界面原文 · 轮次日志面板 轮次 {round_no} 日志 | 自动刷新 | 共 N 条

如果实时连接断了,日志面板会显示一个标签「实时连接已断开,使用轮询」,然后自动改用轮询刷新——不影响你看日志,只是刷新没那么"丝滑"。

3.5 单轮时限:2 小时的"熔断保险丝"

每个任务有一个"时限"字段,默认 7200 秒(2 小时)。这是单轮执行的兜底:万一 AI 卡进死循环或某个外部接口一直不返回,超过时限进程会被强制结束,不会让一轮无限跑下去、把钱和时间都烧光。

你可以按任务复杂度调整它:简单的信息汇总给个 600~1800 秒就够;跑大型代码构建的,给到 7200 秒甚至更长。

3.6 日志面板:想看某次执行到底聊了啥

自动运营控制台 › 日志面板

如果说"运行轮次"是总览,那"日志面板"就是放大镜。它的表格列有:任务 / 轮次 / 状态 / 日志文件 / 更新时间。状态只有两种:运行中(对应正在执行的)和已结束。如果还没有任何日志,空态会提示「暂无日志绑定(任务开始执行后自动生成)」。

点开某一条,就能看这次执行的完整对话记录,面板标题是:

界面原文 · 日志面板标题 任务 {task_id} · 轮次 {round_id} 日志 | 自动刷新

日志会按"项目 → 任务 → 轮次"的顺序组织,你可以顺着往下钻,看 AI 每一步在想什么、调了什么工具、拿到了什么结果。日志支持实时推送和断线重连,刷新是自动的——你不用手动狂点刷新键。

排查问题先看日志

当某个任务反复失败、或验收总是不通过时,最有用的动作不是反复重启,而是打开日志面板,看 AI 最后一次执行卡在哪一步。多半能一眼看出是"外部接口挂了"还是"任务本身描述有歧义"。

四、review 轮:让 AI 抬头看全局,重排任务

如果工厂只会闷头干表上排好的活,早晚会出问题:环境变了、客户需求变了、某件事其实早该停了……所以这套机制安排了一个"定期复盘"的动作,叫 review 轮。

4.1 什么时候会自动触发 review

满足下面任意一条,系统就会插入一轮 review:

触发条件说明
间隔触发距上次 review 已经过了 20 轮(默认值,可配置)
全完成强制触发所有任务都已完成,强制做一次 review 决定下一步
手动触发你主动要求立刻重排(见 4.3)

注意:如果项目正处在"空闲等待"模式(没有未完成任务),系统会忽略"全完成"这条触发,避免陷入"空转→review→还是空→再 review"的死循环。

4.2 review 轮里 AI 到底在看什么

到点后,AI 会"抬头"审视全局,看的东西包括:

然后,它会产出一份"新的排班方案"——重新排布任务集和它们占用的时间片。这份方案会被系统校验后才生效;校验不通过就丢弃重来,不会把乱掉的排班写进去。

4.3 手动触发 review

大多数情况下,AI 会按节奏自动 review。但有时你刚补了需求、或想立刻重排,就可以主动触发一次。

手动触发 review,现在有按钮了

在运行轮次页和自动运营控制台上,都补上了「触发 review」按钮:点一下,系统会在当前轮跑完后插入一次 review 重排。项目里的 AI 对话同样有效(用自然语言说"帮我重排一下任务"),两条路都通。这也对上了第 2.5 节那条空闲等待消息里提示的"触发 review 重排任务"。以实际界面为准。

4.4 review 也会失败,而且有兜底

review 轮本身也可能失败(比如 AI 输出的方案格式不对、模型调用出错)。系统会记一个"review 连续失败计数",处理方式和任务失败一样:连续失败达上限(默认 3 次)就告警并暂停项目循环,等人工介入。这是防烧钱的一环,不要把它当成 bug。

review 成功后,失败会"清零"

失败计数是连续计数:只要有一次 review 成功,之前的失败记录就归零了。所以偶发的失败不会累积成"误熔断"。

五、空闲等待(free):没活干时,别空转烧钱

工厂没订单时,聪明的做法是关灯待工,而不是让机器空转。这套机制也是这样——当没有未完成任务(任务都完成了,或任务集为空)时,项目进入空闲等待模式。

5.1 进入空闲等待后会看到什么

此时系统只做常规检查,不再每一轮都调用 AI。当空闲累计到一定轮数,你会收到一条通知,原文是:

界面原文 · 空闲等待通知 项目已完成全部任务并空闲等待 N 轮(不再消耗 LLM)。如需继续运营,请注入新信息并触发 review 重排任务

在「运行轮次」页,你能看到这些轮次的模式显示为 free。

5.2 "不再消耗 LLM"是什么意思

意思是:空闲等待期间,系统不会逐轮去调模型,因此几乎不产生 token 费用。这对新手特别友好——任务做完了忘了管,也不会默默地一直烧钱。

它会自己"补货",但间隔很大

空闲累计到 10 轮、20 轮、30 轮……这些节点时,系统会尝试让 AI 自己拆解出一批新任务(这叫"AI 补货")。成功拆出新任务,项目就自动退出空闲、继续开工;没拆出来,就继续待工、下个节点再试。所以"空闲"不等于项目死了,只是它暂时没活干。

5.3 怎么把项目从空闲状态"唤醒"

通知里其实已经把答案告诉你了,两步:

  1. 注入新信息:在「任务管理」里新建任务,或编辑已有任务补充新要求(见 2.5);
  2. 触发 review 重排:让 AI 重新看一遍任务集,规划出未完成任务,从而退出空闲模式。
只"注入"不"触发",可能还在待工

光加任务有时还不够——项目的 free 状态是"按任务集重算"的,需要有未完成任务才能退出。最稳的组合是:补任务 + 让它重排一次。如果补了任务后长时间还没动静,就主动触发一次 review。

六、验收:三权分立,谁也不能自审自批

AI 说"我干完了",到底能不能算数?这套机制给出的答案很硬核:不能自审自批。干活的一拨、验收的一拨、批准的一拨,三方分开,这就是三权分立验收。

6.1 一次验收的完整流程

任务输出末尾出现
[Task finished]
→
独立验收 Agent
对照标准评审
→
通过 pass
(标完成)
返工 redo
(重做)
驳回 reject
(升级人工)

验收 Agent 的角色,是独立于执行者的——同一件事不会由干活的 AI 自己打分。它评审的依据,就是你写进任务描述里的"什么算做完"。

6.2 验收的三种结论

结论英文含义与后果
通过pass认定达到标准,任务标记为完成
返工redo没达标,退回让 AI 重做(会累计返工次数)
驳回reject问题较严重,升级到人工处理

返工和驳回都不会无限循环:系统对"驳回"设有上限(默认 3 次),达到阈值就升级人工,防止 AI 在一件事上反复重跑、猛烧钱。

6.3 验收记录页:每一笔验收都留痕

自动运营控制台 › 验收记录

页面标题「验收记录」,顶部可按验收结论(通过 / 返工 / 驳回)、人工状态(待审批 / 已批准 / 已拒绝)、以及任务 ID筛选。

表格列有:验收 ID / 任务 / 结论 / 评分 / 报告 / 人工状态 / 抽样 / 成本 / 时间 / 操作。点「详情」会打开「验收详情」窗口,里面有:验收 ID、任务 ID、执行者、验收 Agent、结论、评分、人工状态、是否抽样、Token 输入、Token 输出、成本,以及三块正文——验收报告、理由(reasons)、证据(evidence_paths)。

"执行者"和"验收 Agent"是两个不同的字段

这正是三权分立的体现:你可以清楚地看到"这活是谁干的"和"这活是谁验的"。如果两个字段指向同一个角色,那就不符合三权分立原则了——不过正常情况下系统会保证它们是分开的。

「抽样」这一列也值得注意:不是每一份产出都会被人工复核,系统会按比例抽样,被抽中的会进入人工审批流程,人工状态随之变为"已批准 / 已拒绝"。

七、人工处理节点:需要你点头的地方

不是所有事都能让 AI 自己拍板。涉及合规风险、花钱、对外发布、删除数据的动作,必须有人参与。这套机制把这些"等人点头"的环节统一成一种东西——人工处理节点。

自动运营控制台 › 人工节点

7.1 三种通道:红黄绿

每个节点都会被系统打上一个"通道"标签,代表它的敏感程度:

绿-例行

例行事项。按自主级别处理,L0 直接执行归档,一般不需要你操心。

黄-敏感

敏感写操作(发布、删除、付费、外发等)。会生成"权限租赁",超权限上限需授权。

红-强制

命中红通道禁止清单。强制 L3 人工审核,AI 不得代行。

7.2 自主级别 L0~L3:AI 能自主到哪一步

项目有一个"自主级别"(默认 L2),它决定了 AI 遇到需要决策的节点时,是"自己干"还是"等你点"。级别从低到高:

级别行为给新手的建议
L0全自主执行,不创建节点、也不通知你只在你非常信任这类事时才用
L1通知不等待:创建节点+通知你,但 AI 继续推进想"知会一声"又不阻塞进度时用
L2(默认)一键确认:AI 暂停等待,你在面板点一下确认才继续推荐。平衡了效率与安全
L3强制人工审核:必须审核通过才继续高风险、合规相关的活

这套级别还有一层"聪明"的地方:系统会按 AI 的历史表现给一个"渐进信任分",分数高就允许更自主(往 L0 靠),分数低就收得更紧(往 L3 靠)。干得好,权限自然放开;干得差,权限自动收紧。

7.3 人工节点页长什么样

页面标题「人工处理节点」,右上角有 新建节点。顶部筛选标签:待处理 / 处理中 / 已完成 / 已驳回 / 已升级。

每个节点以卡片展示,卡片上有:通道、自主级别(L…)、SLA(秒)、处理人、描述。可用的操作按钮是:

按钮作用
确认完成批准这个节点,AI 继续
通知催促重新发一次通知(界面会提示"节点已确认完成/已发送通知"等结果)
升级处理把节点往上抬一级,交给更上级处理
移动审批跳到移动审批页面去处理

7.4 手动建一个节点时填什么

点「新建节点」,弹窗的字段有:标题(必填,如 如:审核营销文案)、描述、自主级别(L0-全自主执行 / L1-通知不等待 / L2-一键确认 / L3-强制人工审核)、关联任务 ID(可选)、SLA 超时(秒)(默认 86400,步进 3600)。

"通道"不在新建表单里

你会发现新建表单里没有"通道"这个字段——因为通道是系统根据动作敏感度自动判定的,你只需要在显示时看它是什么颜色就行,不需要(也不能)手动指定。

7.5 SLA 与双签:节点也会"超时"和"双重把关"

每个节点都有一个 SLA(处理时限)。超过时限没处理,系统会有两种处理方式:配置了"超时降级"的,就降为 L1"通知不等待"、让循环继续;没配置的,就按"升级链"逐级往上找负责人(项目负责人 → 平台超管)。升级链也用尽时,节点会保持挂起——它不会自动放行敏感动作,只是安静地等着人。

对高风险节点(合规、红通道),系统默认要求双签复核(也就是"四眼原则"):需要两位不同的复核人依次确认。第一位确认后节点仍是待处理状态,会去通知第二位;两位都批了才算完成。同一个人没法"双签",任一复核人拒绝,节点即被驳回。

7.6 权限租赁:临时的"放行条"

黄通道的敏感动作,可以申请一张临时的"放行条",即权限租赁。它绑定三样东西:动作(做什么)、到期时间(有效到什么时候)、成本上限(最多花多少钱)。到期或花钱超限就自动回收;执行前系统会检查这张条子还有没有效。

控制台里有一个 权限租赁 快捷入口,可以查看和吊销这些放行条。

八、失败与中断:出问题时,系统怎么刹车

再好的工厂也会出故障。区别在于:好的系统出问题时能安全地停下来,而不是一路烧钱到天亮。这一节讲三道刹车。

8.1 第一道刹车:连续失败的三级兜底

同一个任务连续失败时,系统不是简单地重试,而是逐级加码:

第 1~2 次失败
降级重试
→
第 3 次失败
升级人工
→
超上限
告警退出
阶段系统做什么
第 1~2 次(降级重试)依次尝试:换引擎 → 换角色版本 → 缩小任务范围。换个思路再试,多半能救回来。
第 3 次(升级)让管理者 AI 复盘,并创建一个人工处理节点通知负责人——该人来拿主意了。
超过上限(默认 3 次)告警退出:发通知 + 暂停项目循环,彻底停手防烧钱。
"降级"不是"变差",是"换个打法"

这里的降级指的是换策略(换个引擎、换个角色版本、把任务范围缩小一点),目的是绕开当前失败的路径,让任务能继续推进,而不是降低质量标准。

8.2 第二道刹车:预算预警与熔断

钱是最硬的约束。系统对预算设了两道线:

  1. 预警线(默认 80%):达到时发预算预警通知,提醒你快到上限了;
  2. 熔断线(超预算):AI 运行预算或总预算任一超限,就暂停循环,并通知"预算耗尽,请补充预算后继续";
  3. 单轮上限(默认 100 元/轮):每个任务可以设一个"单轮最大预算"。轮末结算时如果这一轮实际花费超过这个上限,系统会告警并暂停项目,防止某一轮"一口气烧掉一大笔"。这是最后一道按"单班"计的保险,和上面按"总额"计的两条线不冲突。

补充预算后,在控制台点「恢复」或「启动」即可继续——系统会自动复核两条预算线并清除熔断标记。

熔断后不补钱,点"恢复"是没用的

如果预算仍然超限,「恢复」会被拒绝(提示"预算已耗尽,请补充预算后继续")。正确的顺序是:先补充预算,再点恢复。

8.3 紧急停止:KillSwitch

万一出现你完全无法控制的情况(比如 AI 正在执行明显危险的动作),系统提供"紧急停止"开关。它的效果等价于「停止」——硬停循环、状态置为已停止。这是一个"红色按钮",用于最极端的情况。

8.4 中断恢复:断了之后怎么接上

项目可能因为各种原因中断:你点了暂停、人工节点超时、预算熔断、服务器重启……恢复时,系统会按"断了多久"区别对待:

中断时长系统怎么做
豁免期内(默认 2 天内)不做 AI 评估,直接"干净续接"——环境大概率没变,接着干就行
超过豁免期先做环境漂移检查(代码有没有改、依赖有没有变、凭据有没有失效、数据库结构有没有动、知识库有没有更新)

漂移检查之后,系统按中断时长分级(小于 7 天 / 7~30 天 / 超过 30 天),给出三种结论之一:

这些评估结论和最终的人工决定都会留痕,方便你日后回看"当时为什么这么处理"。

为什么"断得越久"越慎重

想象你出差两周回来,桌上那份工作计划的背景可能已经变了:客户换了需求、代码被别人改过、某个 API Key 过期了。中断越久,这些"环境漂移"的概率越高,所以系统要先检查、再决定是"照旧干"还是"重新规划"。

8.5 收尾:终止项目与结项报告

当项目真正做完(或你决定不再做了),点控制台的 终止项目 并填写原因,系统会置为终止态,并自动生成一份结项报告。你也可以随时通过 结项报告 快捷入口查看最近一份。

结项报告通常包含五块内容:目标达成情况、任务完成与返工率、花费与收益、知识沉淀、经验总结。它是做阶段性复盘、或向投资人/老板汇报项目成果时最好用的一份材料。

终止不可逆

终止之后项目就进入终态了,不会再有新的自动运营轮次。所以点它之前,先确认"这个项目确实告一段落了"。如果只是想让它歇一歇,用「暂停」或「停止」,不要用「终止」。

另外还有一个 测试运行 入口,用来查看任务的自检式测试记录(测试 ID、任务、是否通过、引擎、改动说明、测试目标、耗时、时间,以及详情里的"输出尾部""错误信息")。它适合在开发类项目里快速确认"这次改动测过了没有"。

九、计费明细:每一分钱花在哪

自动运营跑起来,钱就像水一样在流。这一页让你把水表看清楚。

自动运营控制台 › 计费明细

9.1 四张汇总卡

累计花费

红色大数字,项目至今花了多少钱。

预算已用

AI 运行预算里已经用掉多少。

输入 Token

累计喂给模型的 token 数量。

输出 Token

累计模型生成的 token 数量。

9.2 计费单价:钱是这么算出来的

AI 的花费,本质上是 token 用量乘以单价。默认单价如下(可在运行配置里调整):

类型默认单价说明
普通输入1 元 / 百万 token含缓存创建部分,统一归入输入
输出2 元 / 百万 token模型生成的部分
缓存读0.02 元 / 百万 token命中缓存的读取,便宜很多

举个例子:输入 100 万 token、输出 50 万 token、缓存读 1000 万 token,总费用约 2.2 元(1×1 + 0.5×2 + 10×0.02)。

有个细节对财务很重要:单价改了,历史流水不会重算。每一笔开销在发生时就按当时的单价"定格"了,后面的调价不影响已经记好的账。

9.3 那两个标签一定要看懂:估算 / 未计量

在"累计花费"卡片旁边,你可能会看到两个小标签。它们是理解这份账单"靠不靠谱"的关键,请务必看清它们各自的官方解释:

界面原文 · 估算标签(悬停可见) 其中包含按文本长度估算的兜底计费(上游未回 usage 时产生),非精确账单,请勿直接作为账单核销
界面原文 · 未计量标签(悬停可见) 这些轮次已实际执行,但没有可用的计量数据(无法读取 usage),仅 0 元留痕,不计入花费
这一页的数字是"运营参考",不是"发票"

"含估算"的部分是按文本长度估出来的,上游没返回用量时才会产生;"未计量"的轮次真的执行了但没读到用量,只按 0 元留痕。所以:不要把这里的数字直接拿去对账或核销。精确账单以平台账本为准。

9.4 按角色、按天看分布

页面下方有两张表,帮你回答"钱被谁花了、哪天花得最多":

页面顶部还有一个"预算消耗"进度条,显示「预算 ¥x / 已用 ¥y」,并用颜色和「已熔断 / 预警」标签提示状态。

十、目标管理:让 AI 干活盯着"目标",而不是"任务清单"

任务是一条条"活",但如果 AI 只盯着任务清单,很容易跑偏——做了一堆活,却没朝你真正想要的方向走。为了解决这个问题,系统引入了一层更高的东西:目标树。

自动运营控制台 › 目标管理

10.1 目标树:愿景 → 目标 → 关键结果 → 任务

它是一棵层级树:最顶层是你的愿景,往下拆成一个个目标,每个目标再拆成若干关键结果(KR),KR 最终挂到具体任务上。这样,每一个任务都知道自己"为了什么"而做。

页面标题「目标管理」,右上角 新建目标。列表里目标的状态有三种:进行中 / 已达成 / 已归档。

10.2 一个目标里都有什么

点开一个目标,能看到:

区块内容
关键结果(KR)每个 KR 有「KR 名称 / 指标 / 目标值 / 当前值」。达成率按各 KR 的权重加权计算。
关联任务这个目标/ KR 下挂着哪些任务(空态显示"暂未关联任务")
权衡权重四项:成本 / 质量 / 风险 / 速度。四项归一化后相加为 1,不填时默认等权(各 0.25)。
升级阈值KR 的加权达成率低于这个阈值时,触发 review 或人工确认。
父目标它在树上的上一级(顶级目标没有父目标)。

10.3 权衡权重:告诉 AI"你更在乎什么"

这四项权重非常实用,是新手最该用起来的一个能力。举个例子:

赶进度的项目:速度 0.4 质量 0.3 成本 0.2 风险 0.1

AI 会更倾向于快速出结果,容忍一定的试错成本。

合规敏感的项目:应把风险的权重调高、成本压低。

如果权重全填成默认等权,AI 可能会为了省钱而承担你不愿承担的风险。

换算成"人话":权重就是你的偏好票。你投给哪一项的权重高,AI 在做取舍时就往那个方向偏。

目标管理的部分能力仍在完善中 部分可用

目标的创建、KR、权重、阈值这些配置和展示是能用的;但"AI 自动把任务拆到 KR 上""任务完成自动回填 KR 进度"这类联动,目前还在推进中。所以现阶段,目标树更多是给你和 AI 一个"共同的靶子",还需要人来对齐。以实际界面为准。

10.4 用对话来管目标

你还可以不点按钮,直接用自然语言在项目对话里驱动管理动作,例如:"帮我新建一个目标:本季度海外询盘量增长 30%""看看现在的目标都达成得怎么样了""把"市场调研"任务的优先级调高一点"。系统内置了一组管理工具,能理解这类指令并落到对应的操作上。写操作(删除、改预算、终止、对外发布)默认会要求人工确认,不会悄悄执行。

十一、日常操作节奏:每天、每周、每月该干什么

机制都懂了,最后落到"你每天实际要动手多久"。给你一份可照做的节奏表。

11.1 每天(5~10 分钟)

11.2 每周(20~30 分钟)

11.3 每月(1~2 小时)

新手最容易忽略的一件事

不是"看数字",而是把任务描述写好。你会发现,凡是返工多、花费高的项目,十有八九是任务描述写得含糊。花十分钟把"什么算做完"写清楚,能省下后面几十上百轮的返工和 token 花费。

11.4 新手最常见的五个误区

误区一:一条大指令干所有事。

把"帮我做营销、发邮件、找客户"塞进一个任务,AI 会不知道从哪下手,验收也没法评。正确做法:拆成"市场调研""写 3 封开发信""发送并跟进"等独立任务。

正解:一个任务对应一件可验收的产出物。

每件产出的"什么算做完"都能一句话说清,验收才有依据。

误区二:所有任务都给高优先级、高权重。

结果就是"人人都是重点=没有重点",紧急的活被摊平,反而更慢。

正解:P0 和高权重留给 1~2 件真正要紧的活。

其余保持 P2、权重 1,让排班表有层次。

误区三:项目卡住了就反复"恢复/启动"。

如果是兜底保护暂停,根因没处理,点了恢复下一轮又被刹停,白折腾。

正解:先看告警原因和日志,处理根因,再恢复。

控制台告警和日志面板,就是给你排查用的。

误区四:把"自动运营"当成"不用管"。

人工节点、验收抽样、预算预警,都需要你定期花几分钟。完全不管,项目迟早卡在某个等你点头的节点上。

正解:每天 5 分钟看一眼,胜过一周后救火。

按 11.1 的四项清单扫一遍即可。

误区五:把计费明细当成精确账单。

里面含"估算"和"未计量"部分,直接拿去对账会出错。

正解:计费明细用来看趋势、做优化,精确账单看平台账本。

两者口径不同,各司其职。

11.5 让 AI 帮你管项目

最后分享一个进阶技巧:这套系统里,很多管理动作都可以用自然语言驱动。你可以在项目对话里直接说,例如:

可直接复制的对话指令 我现在的项目进度怎么样?有哪些任务卡住了?
把"市场调研"任务的优先级调到 P0,权重调到 3。
帮我触发一次 review,重新排一下任务。
最近一周 AI 花了多少钱?哪个角色花得最多?
有哪些人工节点在等我处理?

系统读到这类指令,会自动落到对应的管理操作上。涉及删除、改预算、终止、对外发布等重大写操作时,默认会先要求你确认,不会擅自执行。

十二、本章小结与下一步

这一章内容很密,我们用一句话把整套机制串起来:给工厂排好班(任务+时间片),让它一轮一轮干(轮次+接力),定期抬头重排(review),没活就待工(空闲等待),干完交给独立质检(验收),遇事等人点头(人工节点),出问题就刹车(兜底+预算熔断),全程记好账(计费)。

核心要点回顾

  1. 控制台是总控室:启动 / 暂停 / 恢复 / 停止 / 终止,四个状态搞清楚;"兜底保护暂停"是持久状态,必须人工处理后手动恢复。
  2. 任务的基本单位是"活":写清描述、写好"什么算做完";权重决定精力分配;要交付软件就用"循环执行"。
  3. 10 个时间片 + 任务接力 = 排班表:每轮干一个格子的活,轮末写交接条,下轮接着干。
  4. review 轮定期重排(默认 20 轮或全完成触发);空闲等待不烧钱,靠"注入新信息 + 触发 review"唤醒。
  5. 验收三权分立:完成靠 `[Task finished]` 标记触发独立验收,结论分通过 / 返工 / 驳回。
  6. 三道刹车:连续失败三级兜底、预算 80% 预警与超限熔断、紧急停止开关。
  7. 计费是运营参考而非发票:看懂"估算 / 未计量"两个标签。

下一步

到这里,你已经能独立地把一个项目"跑起来"并"管起来"了。但项目里那些真正复杂的活——比如开发一个新功能、修改一个已有的软件工程——还有一套专门的正道。下一章我们讲:

第10章 软件功能的开发与修改 →

你会看到"软件工程向导"的七个步骤、"软件修改"弹窗怎么用,以及如何用"新建任务"这个正确姿势给项目加功能。

附录 A · 任务描述模板全集

下面 14 条模板,覆盖了新手最常遇到的任务类型。用法:用方括号里的内容替换成你的项目实际信息,直接粘进「任务描述」。每条都包含"什么算做完",这正是 AI 判断是否达标的依据。

A-1 市场调研 调研【目标国家/行业】的【产品/服务】市场:收集至少 15 个有效信息源,覆盖市场规模、主流定价、主要 3~5 个竞品、客户常见痛点。产出结构化报告(含来源链接),每个结论标注信息来源。完成后在末尾标记 [Task finished]。
A-2 竞品分析 分析【竞品名称/网址】:从产品功能、定价策略、目标客户、营销渠道、优劣势五个维度各写一段。产出对比表格 + 3 条"我们可以差异化切入"的建议。信息需来自公开可访问的页面,标注抓取日期。
A-3 营销文案(B2B 邮件) 为目标客户【客户画像】撰写 3 封英文 B2B 开发信:每封含主题行、开场、价值主张、CTA、署名。语言正式、简洁、不夸大承诺;不得出现"AI 生成"字样;发件形象为 ZY Pan。产出后自检拼写与事实。
A-4 内容创作(博客/公众号) 围绕选题【选题】撰写一篇【字数】字的文章:结构为"痛点引入 → 3 个要点 → 实操建议 → 行动号召";给出 3 个备选标题;全文口语化、可读性强。附带 5 条可直接用于社媒的金句。
A-5 数据整理与清洗 把【数据来源/文件】整理为标准表格:字段为【字段1、字段2、…】;处理缺失值、统一日期与金额格式、去除重复行。产出清洗后的文件 + 一份"清洗说明"(记录做了哪些处理、影响了多少行)。
A-6 经营分析报告 基于项目账本与任务数据,产出本【周/月】经营分析报告:包含收入、支出、AI 花费、任务完成率、返工率、环比变化、主要问题与 3 条改进建议。所有数字来自系统真实数据,不估算、不编造。
A-7 客户跟进 针对客户【客户名称】的当前进展【进展描述】,撰写一封跟进邮件:回顾上次沟通要点、给出下一步明确安排、附上所需资料。语气专业友好,英文(海外客户),末尾给出建议跟进时间。
A-8 会议纪要整理 把【会议记录/录音转写】整理成纪要:议题、结论、待办事项(含负责人与截止日期)、遗留问题。待办事项用清单呈现,每项都写明"谁、做什么、什么时候"。
A-9 网站页面文案 为【页面类型:首页/落地页/定价页】撰写文案:包含主标题、副标题、3~4 个卖点模块(每个含小标题与说明)、FAQ 3 条、CTA 按钮文案。面向【目标读者】,突出【核心价值】。
A-10 产品需求梳理 把【原始想法/用户反馈】梳理成需求文档:用户故事(作为…我希望…以便…)、验收标准(每条可验证)、优先级、不做清单(明确写出本次不包含什么)。产出后逐条自检"这条标准能不能验证"。
A-11 知识库入库 把【资料名称】整理为知识库条目:提取关键概念并逐条给出简明定义,标注来源与适用场景,去除过时信息。产出为分节的 Markdown,末尾附"更新记录"。
A-12 定价方案设计 为【产品】设计三档定价:每档写明目标客户、包含功能、价格(含/不含税)、与竞品的相对位置。给出成本底线与毛利率测算,并说明为什么这样分档。所有价格单位统一,标注币种。
A-13 故障排查 排查【现象描述】的问题:列出可能原因并按概率排序,逐条给出验证方法;确认根因后给出修复步骤与回滚方案。产出排查记录(现象 → 假设 → 验证 → 结论 → 修复)。
A-14 周报汇总 汇总本【周】进展:(1)已完成事项及产出物;(2)进行中事项及预计完成时间;(3)遇到的风险与需要的支持。数据来自任务与轮次记录,用事实说话,不写空话。

附录 B · 状态与术语全表

B-1 任务状态

值界面中文含义
pending待执行已登记,等排班轮到它
running运行中正在执行中
paused已暂停被手动暂停,不再被调度
done已完成验收通过
failed失败执行失败,进入兜底流程
planning规划中软件工程/软件修改类任务还在前期规划

B-2 轮次状态

值界面中文
pending待执行
running运行中
passed已通过
redo需重做
rejected已驳回
failed失败

B-3 轮次模式

值中文在干什么
task任务轮正常干一个时间片的活
reviewreview 轮重排任务与时间片
free空闲等待轮没活干,待工省电

B-4 验收结论 / 人工状态

类别值 → 中文
验收结论pass → 通过;redo → 返工;reject → 驳回
人工状态pending → 待审批;approved → 已批准;rejected → 已拒绝
人工节点待处理 / 处理中 / 已完成 / 已驳回 / 已升级
通道red → 红-强制;yellow → 黄-敏感;green → 绿-例行
自主级别L0 全自主 / L1 通知不等待 / L2 一键确认 / L3 强制人工审核
运行模式full_auto → 全自动;semi_auto → 半自动;manual_review → 人工审核
目标状态进行中 / 已达成 / 已归档
引擎loop → 循环执行;agent → Agent 智能体
任务类型general → 通用;eng → 软件工程;mod → 软件修改

B-5 术语人话对照

你可能会听到人话解释
自动运营 / auto-opsAI 自己排班干活的那套机制
轮次 / roundAI 的"一上班",一轮处理一个时间片的活
时间片 / 时间片权重排班表上的格子;权重决定这个任务每轮能占几个格子(精力比例)
任务接力每轮末写一张交接条,下轮接着干
review 轮让 AI 抬头看全局、重排任务
空闲等待 / free没活干时待工省电,不逐轮烧 token
三权分立验收干活的、验收的、批准的不是同一个 AI
人工处理节点需要你点一下才能继续的节点
三通道 red/yellow/green强制人工 / 敏感需确认 / 例行通知
自主级别 L0–L3越高级别 AI 越自由,L2 是默认(需一键确认)
渐进式信任按 AI 的历史表现逐步放开或收紧权限
兜底保护出异常时自动刹车防烧钱的保险
熔断预算超限,循环被自动暂停
KillSwitch紧急停止的红色按钮
权限租赁给敏感动作开的临时"放行条",绑定动作、到期时间、成本上限
环境漂移中断期间代码/依赖/凭据/数据库/知识库发生的变化

附录 C · 排班调度 20 问

1. 我的项目启动了但一直没动静,怎么排查?

按顺序查三件事:①运行模式是不是「全自动」或「半自动」("人工审核"不会自动跑);②自动运营是否已启用;③控制台有没有"兜底保护暂停"告警。三者都正常,再看「任务管理」里有没有任务——没有任务自然没活干。

2. 什么是"时间片"?我要自己去分配吗?

时间片就是排班表上的 10 个格子,系统自动分配,你不用手动排。你要做的只是给任务设"时间片权重"(1~10),决定它占几个格子。权重越高,轮到它的频率越高。

3. 权重设 10 会怎样?会不会把别的任务饿死?

权重 10 的任务几乎每轮都在跑,其它任务的轮次会明显减少。所以别给所有任务都设高权重——那样等于没设。把高权重留给真正紧急重要的 1~2 件活。

4. 任务多了会不会有任务永远轮不到?

不会。未完成任务的权重总和超过 10 时,系统会自动扩容时间片,保证每个任务都能被排上。

5. AI 说干完了,但我觉得没做完,怎么办?

多半是"什么算做完"没写清楚。把任务描述改具体(参考附录 A 的模板),然后触发一次 review 重排。系统也有独立验收 Agent 会把关,验收不通过会退回返工。

6. `[Task finished]` 是什么?我能自己写吗?

它是 AI 在输出末尾打出的"完成标记",系统检测到它才会触发验收。你不需要(也不该)手写它——它是给系统看的信号。你要做的是把"达标标准"写进描述,让 AI 判断何时该打这个标记。

7. review 轮什么时候来?我能要求它立刻来吗?

默认每 20 轮来一次,或所有任务完成时强制来一次。想立刻来,点运行轮次页或自动运营控制台上的「触发 review」按钮即可;在项目对话里说"帮我重排一下任务"同样有效。

8. AI 会不会把我不想删的任务删掉?

review 重排时 AI 确实会重新给出任务集。为了安全,系统会对它产出的排班做校验,不合规的取值会被纠正或丢弃重来。但"少列出一个任务"这种做法,本质上是把该任务移出排班——如果你发现重要的任务莫名消失了,把描述写得更明确、或给它固定更高的权重,并从「任务管理」重新添加。

9. 项目一直在"空闲等待",怎么让它继续干活?

两步:①注入新信息(新建任务或编辑任务补充要求);②触发一次 review 重排。只加任务不重排,有时它还在待工。

10. 空闲等待会一直烧钱吗?

不会。空闲期间不逐轮调模型,通知原文就写着"不再消耗 LLM"。它只在每 10 轮这些节点上尝试"AI 补货"拆新任务,频率很低。

11. 暂停和停止有什么区别?我该用哪个?

暂停是"歇一会儿",当前轮跑完进入等待,随时能「恢复」;停止是"收工",连服务重启都不自动拉起。临时改动用暂停,长期不跑用停止。

12. 为什么暂停后当前这一步还在跑?

这是故意的。暂停不会强杀正在执行的子进程,避免丢掉它已经积累的上下文。等这一轮自然结束,它才进入等待。

13. 项目因为"兜底保护"暂停了,点恢复为什么没用?

兜底暂停是持久状态,光点恢复可能下一轮又被刹停。正确做法:先去"运行配置 / 任务面板"处理掉触发兜底的原因(连续失败、预算超限等),再点「恢复」。注意此时顶部状态标签显示的是「已暂停(兜底)」,不要看到它还挂着"运行中"就以为没事。

14. 连续失败几次会停?

同一任务第 1~2 次失败会降级重试(换引擎→换角色版本→缩小范围),第 3 次升级到人工,超过上限(默认 3 次)就告警并暂停循环。review 轮连续失败同理。

15. 预算到多少会预警?超了会怎样?

默认在 80% 预警;超预算就熔断暂停,并通知你补充预算。补完钱后在控制台点「恢复」或「启动」即可,系统会自动清熔断标记。

16. 中断很久之后再恢复,会不会接不上?

豁免期(默认 2 天)内是"干净续接";超过豁免期,系统会先做环境漂移检查、按时长分级,给出"直接续接 / 调整后续接 / 重新规划"三种结论之一。

17. 计费明细里的钱和实际账单对得上吗?

不一定完全对得上。里面有"按文本长度估算"的兜底部分和"未计量"的轮次,所以这一页是运营参考,不要当发票核销。精确账单以平台账本为准。

18. 单价改了,之前的花费会重算吗?

不会。每笔开销在发生时按当时单价"定格",后续调价不追溯历史。

19. 我点了"人工审核"模式,任务为什么不动了?

因为"人工审核"不启用自动运营循环,任务需要你手动审核/触发才执行。想让它自动跑,切回"全自动"或"半自动"。

20. 目标管理里的"权衡权重"怎么填才对?

四项相加为 1,按你在乎的程度分配。不填时默认等权(各 0.25)。赶进度就抬"速度",重合规就抬"风险",控成本就抬"成本"。它决定了 AI 遇到取舍时往哪边偏。

附录 D · 成本优化清单(15 条)

  1. 把"什么算做完"写进任务描述。这是最省钱的一条——含糊描述导致的返工,是最贵的浪费。
  2. 给任务设合理的时限。简单任务别用默认的 7200 秒,600~1800 秒往往够用,能早点掐掉跑飞的轮次。
  3. 短活优先用 Agent 引擎。信息整合、接口调用、快速查询,用 Agent 比用循环执行省得多。
  4. 权重别乱给高分。只有真正重要的 1~2 个任务配高权重,其余保持低权重,避免"精力均摊"变成"精力浪费"。
  5. 把长任务拆小。一个"边做边验收"的拆解,比一个漫长的巨任务更省钱:早了结、早止损。
  6. 定期看"按角色花费分布"。找出最费钱的角色,优化它的提示词或改用更省的模型。
  7. 把重复性的活固化成模板。提示词模板固定后,AI 不用每次"重新理解需求",token 消耗会明显下降。
  8. 善用缓存。缓存读的单价只有普通输入的 1/50。稳定的上下文更容易命中缓存。
  9. 不要把项目晾在"运行中"却没事干。任务做完就让它进入空闲等待,而不是让它在 task 轮里反复空转。
  10. 及时处理人工节点。节点长时间挂起会拖慢进度、拉长项目周期,间接推高总成本。
  11. 预算预警一响就评估。到 80% 时看一眼"按天分布",判断是该补钱还是该收一收。
  12. 给预算科目分好类。把 token、第三方接口、算力分开记账,才知道钱到底花在哪一类上。
  13. 降低失败率。每一次连续失败都会走到"降级→升级",多花好几轮钱。稳定的外部接口和凭据能省不少。
  14. 不要给不重要的任务配高优先级。P0 会挤占其他人的排班,把紧急留给真紧急。
  15. 阶段性归档已完成目标。目标树保持干净,AI 的每次 review 都会更快、更省钱。

附录 E · 设计依据摘录

本手册的机制描述,来自以下几份正式文档;写"为什么这么设计"时可直接引用。它们也是产品后续演进的方向依据。

主题依据文档关键点
调度与轮次auto-ops 调度与轮次(分卷 04)时间片 + 轮次制;默认 10 个时间片;review 默认 20 轮;单轮默认 7200 秒;接力与完成标记
日志 / 人工 / 预算 / 时限auto-ops 日志人工预算时限(分卷 05)L0–L3 自主级别;红黄绿三通道;双签复核;SLA 升级链;预算 80% 预警、超限熔断;豁免期默认 2 天
分析 / 对话 / 目标 / 计费auto-ops 分析对话目标治理与计费(分卷 06)token 单价(输入 1 元/M、输出 2 元/M、缓存读 0.02 元/M);目标树 KR 加权达成率;权衡权重归一化
接口契约autoops 调度与轮次 API 文档、autoops 人工预算与审计 API 文档生命周期、任务、轮次、human-tasks、budget/state、billing 等端点的字段与语义
关于"已上线 / 部分可用 / 规划中"

本手册用三种标签标注能力现状:已上线 表示前后端都能用;部分可用 表示后端有、界面入口弱或需特定条件;规划中 表示设计在案、尚未开发。你在实际界面看到的功能,以界面为准。